Objectifs d'apprentissage
- Décrire le cycle de vie de pré-entraînement et de réglage fin des LLMs.
- Explorer l'apprentissage par renforcement à partir du retour humain (RLHF).
- Mettre en pratique l'ingénierie de prompt et les méthodes de réglage fin économes en paramètres (PEFT/LoRA).